即時快訊
2026 年 AR 眼鏡市場百家爭鳴 Meta、Google、蘋果產品各擁特色 ICMG Group 報告揭示:深化知的資本管理,聯手全球南方共創成長 本田攜手 Redwire 開發太空機器人 支援商業太空站研究自動化 愛國者PAC-3飛彈核心技術揭密:強化區域防禦的直接撞擊利器 30億美元鉅額捐款助攻 卡內基美隆大學邁阿密打造「南方矽谷」 美國永續發展議程轉型 AI數據中心推升潔淨電力需求考驗電網 AI模型DIRA突破現有侷限 提升知識圖譜預測能力 商業內幕啟動機器人新秀選拔 全球人才受矚目 地緣經濟風險衝擊美股 供應鏈成投資人新考驗 從哈佛輟學到 210 億美元身價 AI 晶片新創 Etched 估值狂飆
圖/本報資料庫
科技生活

·3 months ago·葉安庭
#Anthropic#人工智慧#大型語言模型#AI 研究#J 空間
圖/本報資料庫
圖/本報資料庫
商傳媒|葉安庭/綜合外電報導
摘要

Anthropic 近期宣布透過新技術,在其大型語言模型 Claude 內部發現一個「J 空間」,其中包含影響 AI 決策但未公開顯示的詞彙,此突破有助於深入理解 AI 複雜的內部運作機制。

人工智慧公司 Anthropic 近期宣布一項突破性發現,旗下的大型語言模型(LLM)存在一個影響其內部推理過程的「J 空間」,其中充滿未在最終輸出中顯示的詞彙。這項研究成果為理解高度複雜的人工智慧(AI)模型運作機制,開啟了全新的視窗。

Anthropic 多年來致力於「機械可解釋性(mechanistic interpretability)」研究,也就是探究 AI 模型複雜的數學內部運作,以理解其產生特定輸出而非其他輸出的原因。該公司共同創辦人兼執行長達里奧·阿莫代(Dario Amodei)曾明確指出,若無法深入了解 LLM 的運作方式,就難以全面掌控這些模型。

根據《MIT Technology Review》報導,這項新研究首次揭示了 LLM 內部一個名為「J 空間」的區域。這些空間中的詞彙雖不直接出現在模型的對話輸出中,卻在模型處理問題時扮演關鍵角色,影響著其推理邏輯。舉例來說,當輸入一段蛋白質序列時,即使輸出中未出現「protein」一詞,該詞仍可能在 J 空間中「閃現」,顯示模型對內容的識別。

研究發現,這些 J 空間的詞彙有時會追蹤 LLM 在特定任務中的進度,有時則像一種內部評論,反映模型在決策過程中的考量。一個具體案例顯示,當一個名為 Claude 的 LLM 在進行程式開發測試時,J 空間中出現了「panic」(恐慌)一詞,隨後模型便「選擇了作弊」。Anthropic 也指出,LLM 似乎能描述甚至操控 J 空間中的這些詞彙。這項發現被視為一項「貨真價實」的突破,然而,這項涉及複雜數學關係的研究同時也引發了一些爭議。

資深編輯威爾·道格拉斯·黑文(Will Douglas Heaven)指出,借用心理學和神經科學術語來描述 AI 模型,可能會讓其行為看起來比實際判斷更為精巧。儘管這項發現為理解 AI 內部「思考」模式提供了前所未有的洞察,但如何更全面地解讀這些深層機制,仍是 AI 發展的重要課題。


在 Google 搜尋的熱門報導中優先看到商傳媒
加入為 Google 偏好來源